Cross-Attention Enables Context-Aware Multimodal Skin Lesion Diagnosis
Cette étude démontre qu'un cadre d'apprentissage profond multimodal utilisant un mécanisme d'attention croisée pour intégrer les métadonnées cliniques aux images dermatoscopiques surpasse les stratégies de fusion conventionnelles et les modèles unimodaux dans le diagnostic des lésions cutanées.